Stepfun
-
輸入tokens/百萬
輸出tokens/百萬
上下文長度
Baidu
zelk12
這是一個使用mergekit工具合併的預訓練語言模型,採用DARE TIES方法融合了多個Gemma3-12B變體模型。
grimjim
MagTie-v1-12B是一個基於DARE TIES算法合併的12B參數語言模型,融合了多個預訓練模型的優勢
本項目使用mergekit和DARE TIES方法合併了soob3123/amoral-gemma3-12B-v2和IlyaGusev/saiga_gemma3_12b兩個模型,旨在提供更強大的語言處理能力。
Tarek07
這是一個基於LLaMa-70B架構的多模型融合實驗項目,採用DARE TIES融合方法,結合了6個不同版本的MO-MODEL模型。
ReadyArt
這是一個基於DARE TIES方法合併的12B參數語言模型,融合了多個預訓練模型,旨在提供強大的文本生成能力。
這是一個基於Gemma-2-9B系列模型通過DARE TIES方法融合的9B參數規模語言模型,融合了多個優化版本的Gemma模型。
這是一個使用mergekit和DARE TIES方法合併的預訓練語言模型,基於多個Gemma-2-9B變體模型融合而成。
這是一個基於Gemma-2-9B系列模型的融合模型,採用DARE TIES方法融合了多個Gemma變體,旨在提升文本生成能力。
這是一個基於Gemma-2-9B系列模型通過DARE TIES方法合併的多模型融合版本,整合了多個Gemma變體的優勢。
TareksTesting
使用 DARE TIES 方法合併的預訓練語言模型,基於 L-BASE-V1 融合多個 MERGE 模型
darkc0de
這是一個基於 Mistral-Small-24B-Instruct-2501 的融合模型,採用了 DARE TIES 融合方法,整合了多個 24B 參數規模的模型。
DavidAU
一個用於創意、頭腦風暴、角色扮演、長篇故事、場景及虛構內容生成的模型,以獨特方式融合多個模型,生成極具創意且不可預測的文本內容。
rmihaylov
基於Meta-Llama-3-8B和Meta-Llama-3-8B-Instruct模型,採用DARE TIES合併方法創建的預訓練語言模型
BioMistral
BioMistral-MedMNX 是一個通過融合多個預訓練模型而創建的生物醫學領域專用語言模型,採用 DARE 和 TIES 融合方法優化性能。
jambroz
這是一個使用mergekit工具通過DARE TIES方法合併的7B參數規模語言模型,融合了多個高性能開源模型。
Natkituwu
Erosumika-7B-v3是一個7.1bpw exl2量化的語言模型,適合在8GB顯存的GPU上運行16k上下文。它是通過DARE TIES方法融合多個模型而成,主要用於娛樂性質的虛構寫作。
sophosympatheia
Midnight Rose是通過DARE TIES方法融合多個70B參數模型而成的創意寫作專用大語言模型,在角色扮演和故事創作方面表現優異。
brucethemoose
這是一個基於Yi-34B-200K基礎模型,通過DARE Ties方法合併多個同源模型的高密度合併模型,具有200K長上下文處理能力。
這是一個通過mergekit的DARE Ties方法合併的34B參數大語言模型,基於Yi-34B-200K架構,融合了Nous-Capybara-34B、Tess-M-v1.3和airoboros-3_1-yi-34b-200k三個模型的能力。